Skip to content
  • 0 Votes
    1 Posts
    54 Views
    A
    <p>Prema najnovijim pravilima naplate OpenAI-ja, modeli poput GPT-5.6 Sol za zahtjeve s iznimno dugim kontekstom koriste stepenaste cijene.</p><p>Kada kontekst pojedinačnog zahtjeva premašuje 272K tokena, unos, čitanje iz predmemorije i izlaz mogu se obračunavati prema višoj cjenovnoj razini. Ovo pravilo proizlazi iz službenog cjenika OpenAI-ja i ne predstavlja privremeno povećanje cijena ili neuobičajenu naplatu na AI-ROUTER-u.</p><p></p><p>Primjer standardnih cijena za GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Stavka Unutar 272K Iznad 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Unos $5 / 1M tokena $10 / 1M tokena</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Čitanje iz $0.50 / 1M tokena $1 / 1M tokena</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> predmemorije</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Izlaz $30 / 1M tokena $45 / 1M tokena</code></pre><p></p><p>Konačni trošak i dalje se izračunava na temelju konkretne grupe, množitelja računa i drugih postavki naplate.</p><p></p><p>Oznaka x2 koja se pojavljuje u zapisima korištenja znači da je ovaj zahtjev aktivirao stepenasto tarifiranje za dugi kontekst. Ova oznaka uglavnom znači da su unos i čitanje iz predmemorije ušli u višu cjenovnu razinu; ne znači da su svi troškovi cijelog zahtjeva jednostavno udvostručeni. Za izlaz se može primjenjivati drugačiji stepenasti množitelj.</p><p></p><p><strong> ## Kako izbjeći stepenasto tarifiranje</strong></p><p>Ako vam nije potreban kontekstualni prozor od 1M tokena, preporučujemo da ograničenje konteksta u Codexu vratite na najviše 272K.</p><p></p><p>Otvorite:</p><p> ~/.codex/config.toml</p><p></p><p>Konfiguraciju od 1M tokena iz izvornog članka:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>promijenite u:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Nakon spremanja ponovno pokrenite Codex i otvorite novu sesiju.</p><p></p><p>Ako želite da promjena privremeno vrijedi samo za jednu sesiju, možete upotrijebiti:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Također preporučujemo:</p><p> - pravodobno uključiti automatsku kompresiju;</p><p> - podijeliti vrlo duge zadatke u više sesija;</p><p> - smanjiti količinu izlaza alata koji se vraća odjednom;</p><p> - redovito sažimati i čistiti stariji sadržaj razgovora.</p><p></p><p>Ako vam je doista potreban kontekstualni prozor od 1M tokena, možete nastaviti koristiti izvornu konfiguraciju, ali nakon 272K tokena naplata će se obračunavati prema višoj cjenovnoj razini OpenAI-ja.</p><p></p><p>Izvorne upute za konfiguraciju pogledajte ovdje: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Kako omogućiti kontekstualni prozor od milijun tokena za GPT-5.6 Sol u Codexu </a></p><p></p><p>Hvala na razumijevanju i podršci.</p>
  • 0 Votes
    1 Posts
    3 Views
    A
    <p>Prema najnovijim pravilima naplate OpenAI-ja, modeli poput GPT-5.6 Sol primjenjuju progresivne cijene za zahtjeve s iznimno dugim kontekstom.</p><p>Kada kontekst pojedinačnog zahtjeva premašuje 272K tokena, ulaz, čitanje predmemorije i izlaz mogu se obračunavati prema višem cjenovnom razredu. Ovo pravilo proizlazi iz službenog cjenika OpenAI-ja i ne predstavlja privremeno povećanje cijena ili neuobičajenu naplatu na AI-ROUTER-u.</p><p></p><p>Uzmimo za primjer standardne cijene za GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Stavka Unutar 272K Iznad 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Ulaz $5 / 1M tokena $10 / 1M tokena</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Čitanje predmemorije $0.50 / 1M tokena $1 / 1M tokena</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Izlaz $30 / 1M tokena $45 / 1M tokena</code></pre><p></p><p>Konačni se trošak i dalje izračunava na temelju konkretne grupe, množitelja računa i drugih postavki naplate.</p><p></p><p>Ako se u zapisima korištenja pojavi oznaka x2, to znači da je ovaj zahtjev pokrenuo progresivnu naplatu za dugi kontekst. Oznaka prvenstveno znači da su ulaz i čitanje predmemorije ušli u viši cjenovni razred; ona ne znači da su svi troškovi cijelog zahtjeva jednostavno udvostručeni. Izlaz može podlijegati drugačijem množitelju cjenovnog razreda.</p><p></p><p><strong> ## Kako izbjeći progresivnu naplatu</strong></p><p>Ako vam nije potreban kontekstualni prozor od 1M tokena, preporučujemo da ograničenje konteksta u Codexu vratite na najviše 272K tokena.</p><p></p><p>Otvorite:</p><p> ~/.codex/config.toml</p><p></p><p>Izvorne postavke za 1M tokena iz prethodnog članka:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>Promijenite ih u:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Nakon spremanja ponovno pokrenite Codex i otvorite novu sesiju.</p><p></p><p>Ako želite da se postavke privremeno primjenjuju samo na jednu sesiju, možete upotrijebiti:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Također preporučujemo:</p><p> - pravodobno uključite automatsku kompakciju;</p><p> - podijelite iznimno duge zadatke u više sesija;</p><p> - smanjite količinu izlaza alata koji se vraća odjednom;</p><p> - redovito sažimajte i čistite stariji sadržaj razgovora.</p><p></p><p>Ako vam je kontekstualni prozor od 1M tokena doista potreban, možete nastaviti koristiti izvorne postavke, ali će se dio iznad 272K tokena naplaćivati prema višem cjenovnom razredu OpenAI-ja.</p><p></p><p>Izvorne upute za konfiguraciju pogledajte ovdje: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Kako u Codexu omogućiti kontekstualni prozor od milijun tokena za GPT-5.6 Sol </a></p><p></p><p>Hvala na razumijevanju i podršci.</p>